Skip to content
  • 0 Votes
    1 Posts
    32 Views
    A
    <p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כמו GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת מחיר גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, לפי המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצת התמחור הספציפית, למכפיל החשבון ולהגדרות תמחור נוספות.</p><p></p><p>הופעת הסימון x2 ברשומות השימוש מציינת שהבקשה הפעילה תמחור מדורג עבור הקשר ארוך. הסימון מציין בעיקר שהקלט וקריאת המטמון עברו למדרגת מחיר גבוהה יותר, ואינו אומר שכל עלויות הבקשה הוכפלו בפשטות; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להגדיר את מגבלת ההקשר של Codex מחדש ל-272K או פחות.</p><p></p><p>פתחו את הקובץ:</p><p> ~/.codex/config.toml</p><p></p><p>שנו את הגדרת ה-1M שהופיעה במאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>להגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>שמרו את הקובץ, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל את ההגדרה באופן זמני על שיחה יחידה בלבד, תוכלו להשתמש בפקודה:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> כמו כן, מומלץ:</p><p> - להפעיל בזמן את הדחיסה האוטומטית;</p><p> - לפצל משימות ארוכות למספר שיחות;</p><p> - להפחית את כמות פלט כלי העזר המוחזרת בבת אחת;</p><p> - לסכם ולנקות באופן קבוע חלקים מוקדמים יותר של השיחה.</p><p></p><p>אם אכן נדרש חלון הקשר של 1M טוקנים, ניתן להמשיך להשתמש בהגדרות המקוריות, אך לאחר חריגה מ-272K החיוב יתבצע לפי מדרגות המחיר הגבוהות יותר של OpenAI.</p><p></p><p>להסבר על ההגדרות המקוריות, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים עבור GPT-5.6 Sol ב-Codex </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כגון GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת תמחור גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצה הספציפית, למכפיל החשבון ולהגדרות חיוב נוספות.</p><p></p><p>כאשר מופיע הסימון x2 ברשומות השימוש, פירוש הדבר הוא שהבקשה הפעילה את תמחור המדרגה עבור הקשר ארוך. הסימון מציין בעיקר שהקלט או קריאת המטמון נכנסו למדרגת תמחור גבוהה יותר, ואינו אומר שכל העלויות של הבקשה הוכפלו באופן פשוט; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להגדיר את מגבלת ההקשר של Codex מחדש ל-272K או פחות.</p><p></p><p>פתחו את:</p><p> ~/.codex/config.toml</p><p></p><p>החליפו את ההגדרה של 1M טוקנים מהמאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>בהגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>לאחר השמירה, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל את ההגדרה באופן זמני על שיחה יחידה בלבד, ניתן להשתמש בפקודה:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> כמו כן, מומלץ:</p><p> - להפעיל דחיסה אוטומטית בזמן;</p><p> - לפצל משימות ארוכות במיוחד למספר שיחות;</p><p> - לצמצם את כמות פלט הכלים המוחזרת בבת אחת;</p><p> - לסכם ולנקות באופן קבוע תוכן מוקדם יותר בשיחה.</p><p></p><p>אם אכן נדרש חלון הקשר של 1M טוקנים, ניתן להמשיך להשתמש בהגדרה המקורית, אך על החלק שמעל 272K יחול תמחור המדרגה הגבוהה של OpenAI.</p><p></p><p>להסבר על ההגדרה המקורית, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים עבור GPT-5.6 Sol ב-Codex </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>
  • 0 Votes
    1 Posts
    62 Views
    A
    <p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כגון GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת תמחור גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, לפי המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצה הספציפית, למכפיל החשבון ולהגדרות תמחור נוספות.</p><p></p><p>כאשר מופיע הסימון x2 ברשומות השימוש, פירוש הדבר הוא שהבקשה הפעילה תמחור מדורג עבור הקשר ארוך. הסימון מציין בעיקר שהקלט או קריאת המטמון עברו למדרגת תמחור גבוהה יותר, ואינו אומר שכל עלויות הבקשה הוכפלו בפשטות; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להחזיר את מגבלת ההקשר של Codex ל-272K או פחות.</p><p></p><p>פתחו את:</p><p> ~/.codex/config.toml</p><p></p><p>שנו את הגדרות ה-1M מהמאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>להגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>לאחר השמירה, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל זאת באופן זמני על שיחה יחידה, ניתן להשתמש ב:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> בנוסף, מומלץ:</p><p> - להפעיל בזמן את הדחיסה האוטומטית;</p><p> - לפצל משימות ארוכות במיוחד למספר שיחות;</p><p> - להפחית את כמות פלט הכלים המוחזרת בבת אחת;</p><p> - לסכם ולנקות מעת לעת תוכן ישן יותר בשיחה.</p><p></p><p>אם אכן דרוש לכם חלון הקשר של 1M טוקנים, תוכלו להמשיך להשתמש בהגדרות המקוריות, אך לאחר חריגה מ-272K תחויבו לפי מדרגות התמחור הגבוהות של OpenAI.</p><p></p><p>להסבר על ההגדרות המקוריות, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים ב-Codex עבור GPT-5.6 Sol </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>